AI资讯新闻榜单内容搜索- Claude Op

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索:  Claude Op
Agent记忆新范式Recuris:3B小模型到Claude Opus 5全线暴涨

Agent记忆新范式Recuris:3B小模型到Claude Opus 5全线暴涨

Agent记忆新范式Recuris:3B小模型到Claude Opus 5全线暴涨

在此背景下,新加坡国立大学、普林斯顿大学与斯坦福、牛津等研究团队合作提出了 Recuris(Recursive Experiential–Working Memory Evolution),作为首个将递归自我改进应用在记忆控制层内的智能体架构,Recuris 通过三项核心技术突破,无需训练即成功实现了从 3B 小模型到 Claude Opus 5 的全面提升。

来自主题: AI技术研报
9399 点击    2026-08-30 11:55
华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。

来自主题: AI技术研报
8516 点击    2026-08-25 14:56
ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维

ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维

ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维

7 月 16 日,伯克利博士后 Haven Feng 的一条推文火了。原因无他,结果很震撼:在 ARC-AGI-3 Public 集上,一套名为 [schema] 的智能体框架,与 Claude Opus 4.8、Fable 5 组合后达到 98.98% 的 RHAE;换成 GPT-5.6 Sol 组合,分数也有 95.35%。

来自主题: AI技术研报
10147 点击    2026-07-18 14:22
刚刚,Mind Lab开源V1系列模型Preview,749B参数,专为Agent 后训练

刚刚,Mind Lab开源V1系列模型Preview,749B参数,专为Agent 后训练

刚刚,Mind Lab开源V1系列模型Preview,749B参数,专为Agent 后训练

过去一个多月,大模型圈依旧热闹。从 GPT-5.5、DeepSeek V4 到 Claude Opus 4.8,后训练正在成为模型能力提升的关键引擎。

来自主题: AI技术研报
9590 点击    2026-06-08 15:29
Claude Opus 4.8蒸馏国产大模型Qwen、DeepSeek,网友晒实锤!

Claude Opus 4.8蒸馏国产大模型Qwen、DeepSeek,网友晒实锤!

Claude Opus 4.8蒸馏国产大模型Qwen、DeepSeek,网友晒实锤!

网上有条帖子炸了,稳定复现,通过 API 问 Claude Opus 4.8 你是什么模型。回答是:Qwen,或者 DeepSeek。重要的事说三遍:必须是通过 API,必须是通过 API,必须是通过 API。因为网页端有系统提示词,会做二次处理。

来自主题: AI资讯
10941 点击    2026-05-29 13:04
Anthropic官宣融资4407亿,估值超越Openai,同时最强通用模型 Claude Opus 4.8 登场

Anthropic官宣融资4407亿,估值超越Openai,同时最强通用模型 Claude Opus 4.8 登场

Anthropic官宣融资4407亿,估值超越Openai,同时最强通用模型 Claude Opus 4.8 登场

Anthropic最强通用模型Claude Opus 4.8正式发布,新模型基准测试全面超越Gemini 3.1 Pro、Opus 4.7,仅一项逊色于GPT-5.5,但其标准模式价格不变,快速模式价格仅为Opus 4.7的1/3。与此同时,Anthropic还官宣一笔650亿美元(约合人民币4406.94亿元)H轮巨额融资,投后估值冲上9650亿美元(约合人民币6.54万亿元)

来自主题: AI资讯
12152 点击    2026-05-29 10:40
DeepSeek、Claude、GPT、Gemini、Qwen实测五大旗舰模型AI编程能力,看Qwen3.7 Max 是否实至名归?!

DeepSeek、Claude、GPT、Gemini、Qwen实测五大旗舰模型AI编程能力,看Qwen3.7 Max 是否实至名归?!

DeepSeek、Claude、GPT、Gemini、Qwen实测五大旗舰模型AI编程能力,看Qwen3.7 Max 是否实至名归?!

超越 GPT-5.5、Gemini 3.5 Flash、DeepSeek V4 Pro,阿里的最新旗舰模型 Qwen3.7 Max 在编程竞技榜拿下第二名,仅次于 Claude Opus 4.7。除了真实场景的用户选择,在传统的大模型固定评测榜单上,像是终端能力 Terminal Bench、编程能力 SWE Bench 等,Qwen3.7 Max 的表现也是拿下了国产模型的冠军。

来自主题: AI产品测评
12801 点击    2026-05-28 12:06
手把手教你免费领 Claude Opus 4.7 + 半价 ChatGPT Plus

手把手教你免费领 Claude Opus 4.7 + 半价 ChatGPT Plus

手把手教你免费领 Claude Opus 4.7 + 半价 ChatGPT Plus

上次给大家写了《Codex教程》之后,评论区里陆陆续续冒出来好多问题。问的最多的,是土区订阅 ChatGPT Plus 的事。既然是已经存在的定价差异,还有那么多人不知道,那就写,写清楚,手把手教到会为止。

来自主题: AI资讯
15412 点击    2026-05-16 11:30
Cursor 上线 Claude Opus 4.7「极速模式」:快 2.5 倍,贵 6 倍,官方劝你别用!

Cursor 上线 Claude Opus 4.7「极速模式」:快 2.5 倍,贵 6 倍,官方劝你别用!

Cursor 上线 Claude Opus 4.7「极速模式」:快 2.5 倍,贵 6 倍,官方劝你别用!

Cursor 正式接入 Claude Opus 4.7 Fast mode——同一个旗舰模型,拆出两个速度档。快 2.5 倍,贵 6 倍,输出价每百万 token 150 美元。最离谱的是,Cursor 官方在发布当天就建议:多数任务请用标准速度。

来自主题: AI资讯
10882 点击    2026-05-14 15:00